Claude Opus 4.6 на Anthropic откри над 500 непознати критични уязвимости в open-source библиотеки

Новият модел Claude Opus 4.6 на Anthropic е открил над 500 неизвестни досега високорискови уязвимости в open-source библиотеки с малко или без конкретни инструкции. Компанията посочва, че всяка уязвимост е била потвърдена от член на екипа на Anthropic или от външен изследовател по сигурността.
Развитието идва на фона на нарастваща надпревара между защитници и атакуващи, при която AI може едновременно да подобри защитата и да увеличи мащаба и сложността на атаките.
Как е тестван Claude Opus 4.6
Преди публичното представяне на Claude Opus 4.6, т.нар. frontier red team на Anthropic е провел тестове в изолирана (sandboxed) среда, за да оцени доколко моделът може да намира дефекти в open-source код.
Екипът е осигурил на модела достъп до Python и инструменти за анализ на уязвимости, включително класически дебъгъри и fuzzing инструменти, но без да му дава конкретни инструкции или специализирани предварителни знания за целевите проекти.
Какви уязвимости са открити
По данни на Anthropic, откритите zero-day уязвимости включват проблеми, които могат да бъдат използвани за срив на системи, както и дефекти, свързани с корупция на паметта.
В публикация в блог компанията дава примери за конкретни проекти:
- GhostScript – популярна програма за обработка на PDF и PostScript файлове; Claude е идентифицирал дефект, който може да доведе до срив.
- OpenSC – инструмент за обработка на данни от смарт карти; открити са уязвимости от тип buffer overflow.
- CGIF – инструмент за обработка на GIF файлове; също са открити проблеми от тип buffer overflow.
Когато традиционните методи не намират нищо
Anthropic описва случаи, в които Claude Opus 4.6 е използвал по-усъвършенствани умения за разсъждение, за да изведе нови подходи за търсене на грешки.
При дефекта в GhostScript моделът е насочил анализа си към историята на Git commit-ите на проекта, след като както fuzzing (подаване на произволни/невалидни входни данни към кода), така и ръчен анализ не са открили проблеми. След установяване на уязвимостта моделът е предприел допълнителни стъпки, за да провери дали подобен проблем не съществува и на други места в кода.
В случая с CGIF Claude дори сам е създал proof-of-concept, за да демонстрира, че уязвимостта е реално експлоатируема.
Контроли срещу злоупотреба и следващи стъпки
Компанията съобщава, че е добавила нови мерки за сигурност към последната версия на Claude Opus, насочени към по-бързо откриване и реакция спрямо опити за злоупотреба с кибер възможностите на модела. Това може да включва инструменти за детекция в реално време, които да блокират трафик, който Anthropic счита за потенциално злонамерен.
Anthropic предупреждава, че подобни мерки вероятно ще създадат допълнително „триене“ и за легитимни изследвания и част от защитните сценарии, затова компанията заявява намерение да работи със общността от security изследователи, за да се намират решения при възникване на проблеми.
Ръководителят на frontier red team на Anthropic Логан Греъм (Logan Graham) посочва, че компанията разглежда начини да направи тези способности за откриване на уязвимости по-достъпни за по-широката общност по киберсигурност, включително чрез потенциални нови инструменти.
Какво означава това
- AI моделите могат да ускорят откриването на zero-day уязвимости в open-source компоненти, които стоят в основата на корпоративен софтуер и критична инфраструктура.
- „Out-of-the-box“ откриването на дефекти подсказва, че защитните екипи могат да получат нов клас инструменти, които допълват fuzzing, дебъгване и ръчен преглед.
- Същите възможности увеличават риска от злоупотреба, което прави контролите за безопасност и мониторинга на използването ключови.
- Въвеждането на по-строги защити може да усложни легитимната изследователска работа, затова ще са нужни механизми за баланс между сигурност и полезност.



